AI资讯新闻榜单内容搜索-Claude

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Claude
「自验证」框架让开源模型反超 Fable 5,冲上 GitHub 热榜

「自验证」框架让开源模型反超 Fable 5,冲上 GitHub 热榜

「自验证」框架让开源模型反超 Fable 5,冲上 GitHub 热榜

随着开源模型能力不断提升,它们已经能够以极低的成本生成多个高质量候选方案,并进一步利用模型自身对这些结果进行验证、打分和筛选。斯坦福团队最新实验发现,使用 DeepSeek V4 Flash + LLM-as-a-Verifier 进行「自验证」,可以在 Terminal-Bench 2.1 上超越 Claude Fable 5,同时整体成本低约 11 倍。

来自主题: AI技术研报
6467 点击    2026-08-28 12:01
刚刚,Claude Code又进化了,替用户起草「反馈报告」

刚刚,Claude Code又进化了,替用户起草「反馈报告」

刚刚,Claude Code又进化了,替用户起草「反馈报告」

Claude Code 又更新了一个颇有意思的小功能。 这一次,它可以帮你起草反馈报告了。 当某个功能出现故障、Claude 发现自己犯了错误,或者你告诉它哪里出了问题时,它会自动把相关情况整理成一份报告。

来自主题: AI资讯
9948 点击    2026-08-27 15:12
全公司禁用Claude Code,CEO放狠话逼宫A社!

全公司禁用Claude Code,CEO放狠话逼宫A社!

全公司禁用Claude Code,CEO放狠话逼宫A社!

因为一份Markdown,Claude Code可能要被踢出门了。最近,Shopify CEO Tobi Lütke突然在X上发话——我正在考虑禁止Shopify使用Claude Code。除非他们改主意,开始支持读取AGENTS.md和.agents/skills 。

来自主题: AI资讯
7922 点击    2026-08-27 09:32
突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌

突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌

突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌

今天,又有消息曝出:全新Opus 5.1模型,据传将在本周突袭发布。 从此,智能体赛道又要大洗牌了。 它有碾压级的编程能力、复杂的逻辑推理和长时间运行的AI Agent能力。单Token的智能水平,将再次被推到极限!

来自主题: AI资讯
9413 点击    2026-08-26 20:24
6个Claude Code神作,Anthropic亲选

6个Claude Code神作,Anthropic亲选

6个Claude Code神作,Anthropic亲选

最近,Claude 官方晒出了不少很酷的 Claude Code 项目。

来自主题: AI资讯
8599 点击    2026-08-25 15:22
华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。

来自主题: AI技术研报
8655 点击    2026-08-25 14:56
一行命令,我把 Claude Code 和 Codex 打通了

一行命令,我把 Claude Code 和 Codex 打通了

一行命令,我把 Claude Code 和 Codex 打通了

关于无缝衔接 Claude Code 和 Codex 这件事。

来自主题: AI技术研报
9482 点击    2026-08-24 16:48
深度|对话 Claude Code 之父:当模型越来越聪明,还在设计复杂工作流的人只是在假装做产品

深度|对话 Claude Code 之父:当模型越来越聪明,还在设计复杂工作流的人只是在假装做产品

深度|对话 Claude Code 之父:当模型越来越聪明,还在设计复杂工作流的人只是在假装做产品

2024 年,Boris Cherny 加入 Anthropic 时,AI 编程产品大多还停留在代码补全和对话问答阶段。模型已经能够写出完整的函数和文件,但产品通常只允许它在编辑器里提出建议,很少真正赋予它读取代码库、修改文件和调用终端的能力。

来自主题: AI资讯
8930 点击    2026-08-24 09:17
首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?

首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?

首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?

Claude Opus 4.6的轻量平替,只需要 27B 参数,你信吗?最近发布的Qwen3.8-27B,就顶着这样的评价火遍了开源社区。上线两天,下载量突破100万次,登顶Hugging Face全球大模型趋势榜。

来自主题: AI产品测评
11511 点击    2026-08-23 14:12